El Concepto Clave: Cerebros y Manos
En nuestros laboratorios anteriores, vimos lo potentes que son los Grandes Modelos de Lenguaje (LLMs, por sus siglas en inglés), pero también identificamos una gran debilidad: están encerrados en una caja. Solo conocen aquello con lo que fueron entrenados y no pueden interactuar con el mundo real.
Los Agentes de IA resuelven este problema combinando dos componentes distintos:
- El Cerebro: El LLM (como Qwen3-4B), que comprende el lenguaje humano, maneja la lógica y mantiene el contexto de la conversación.
- Las Manos: Código Python y herramientas externas (APIs) que pueden interactuar activamente con el mundo real, como consultar el clima, navegar por internet o realizar cálculos.
Enseñando al Cerebro a Usar las Manos
Un LLM no puede "hacer clic" en botones ni "ejecutar" Python de forma natural. Hoy, nuestro objetivo es enseñar al Cerebro a reconocer cuándo necesita ayuda y a formatear su salida para que nuestro programa Python pueda ejecutar la herramienta por él.
